在航天装备高密度发射形势下,软件作为各类系统产品的“神经中枢”,其规模呈指数级增长,且逻辑复杂度日益攀升。面对海量代码与紧迫周期的双重挑战,中国航天科技集团有限公司八院804所软件测评中心以“领域知识库+专家大模型+行业智能体”三维一体的数智赋能技术路线,开发软件智能测试系统,推动软件测评模式转型。
破局之道,在于“智”变
航天任务复杂度指数级增长和软件快速迭代使传统软件测评模式“捉襟见肘”。文档编写耗时费力、用例覆盖存在盲区、代码走查过度依赖经验……这些“人工依赖”的痛点,正成为制约型号任务高效推进的瓶颈。
“人工智能大模型的出现使软件研制开发的流程重塑成为可能,这也是适应当前形势的必然要求。”软件测评中心负责人于清华说。
测评中心立足20余年测评数据积淀,基于“大模型+小模型”协同、检索增强生成技术与智能体自主决策的深度融合,将海量历史测评数据、典型问题、测试标准等内容进行结构化存储,为大模型提供优质的数据基座,构建起一套覆盖测评全生命周期的智能化闭环体系,推动软件质量保障从“经验驱动”向“数据与算法驱动”转型。
持续升级,焕发新生
“过去,编写一份测试大纲、梳理一套用例,往往需要耗费数天时间,且难免出现疏漏。现在,软件智能测试系统成了测评人员非常得力的帮手。”中心副主任高赛军介绍。
针对测评文档编写痛点,测评中心创新构建了测评设计智能生成系统。依托筛选后的高质量历史知识库,系统能够理解需求文档,自动拆解任务,驱动智能体生成测试大纲、测试用例及测试报告。测评人员从此得以解放出来,将精力聚焦于更具创造性的测试策略设计与质量分析。
得益于大量智能工具的集成,该系统的应用场景不仅涵盖文档处理、图片处理等基本任务,还能迭代出代码缺陷智能检测等升级功能。此外,系统还内嵌可全面评估任务全过程的反馈评价机制,在使用过程中通过分析智能体在任务过程中的每一步行动,精确定位性能瓶颈,为智能体提供持续改进的反馈信息,形成评估与优化的闭环,持续赋能测评效率与质量双提升。
体系赋能,构建防线
智能软件在航天领域的应用逐渐普及,但同时也带来了新的测评难题,构建新型评估体系、建立智能软件质量的“标尺”被提上日程。
构建智能软件测试体系,一方面可以实现测试能力提升,另一方面还可通过完善智能软件测试流程、制定智能软件测试标准,逐步推动智能软件评估体系标准化。目前该系统已应用于多项智能系统的测试评估,能够发现多类传统测试模式中难以察觉的问题,对于提升智能系统的可靠性起到了很大的作用。
今年以来,随着数智赋能平台的试点验证与迭代优化,804所智能测试逐步落地。从新型算力底座的强力支撑,到强悍大模型的深度集成,再到自主可控的算法架构,804所正在软件智能化测试领域迈出坚实的步伐。
(邓一帆 薛漭潮)